
為符合歐洲聯盟《AI法案》的最新規定,OpenAI 已在其AI模型 ChatGPT 和 Codex 於歐盟地區生成的文字內容中導入隱形浮水印,這項技術能在不影響閱讀下追溯AI生成痕跡,但OpenAI也提醒大幅修改可能影響偵測。
為因應歐盟《人工智慧法案》(AI Act)對AI生成內容透明度的要求,OpenAI宣布將在未來數週內,逐步為歐盟地區符合條件的ChatGPT與Codex文字輸出加入不可見的文字浮水印,協助外部系統辨識內容是否可能由OpenAI模型生成。
這項名為「textGrain」的技術並非在文字中加入肉眼看不到的特殊字元、空格或符號,而是微幅調整模型生成文字時的選字機率,在整段內容中形成特定統計模式。經由專用偵測工具分析後,即可判斷文字是否帶有OpenAI的浮水印訊號。
OpenAI表示,這項措施主要回應歐盟AI法案對生成式AI內容的可識別性要求。相關規範要求AI生成或修改的內容應以機器可讀方式標記,讓平台、研究人員或其他系統有機會辨識其來源,提高AI內容透明度。
不過,文字浮水印並非百分之百可靠。OpenAI指出,短篇文字、格式限制較高的內容,以及經過大量改寫、重新措辭或翻譯後的文字,都可能降低偵測準確度;偵測系統也可能出現誤判或未能辨識的情況。因此,即使沒有偵測到浮水印,也不能直接證明內容一定由真人撰寫。
另一方面,即使成功偵測到浮水印,也只能代表文字可能曾由OpenAI系統生成或處理,無法進一步判斷使用者身分、人工參與程度、內容所有權,或文字本身是否正確。因此,浮水印較適合作為內容來源的輔助訊號,而不是判斷真偽的唯一依據。
目前OpenAI規劃先在歐盟地區的ChatGPT與Codex逐步啟用文字浮水印,全球API客戶則可自行選擇是否啟用部分模型的文字浮水印功能,預設仍為關閉。公司也將開放部分經核准的研究機構及專業組織使用偵測工具,以進一步評估技術表現。
對歐洲企業而言,這項變化意味著AI內容管理將進一步納入合規流程。企業若使用ChatGPT或Codex協助撰寫文件、內容製作或其他文字工作,未來除了關注資料隱私、著作權與內部AI使用規範,也可能需要考量生成內容的標示與可追溯性。
整體而言,隨著歐盟AI法案透明度規範逐步落實,AI生成內容的來源辨識正從圖片與影音進一步延伸至文字。OpenAI此次導入textGrain,也反映生成式AI業者正加速建立內容溯源機制,但相關技術仍有侷限,未來如何在辨識效果、使用便利性與隱私之間取得平衡,仍將是AI治理的重要議題。
